「反正寫完會跑掃描工具檢查,動筆的時候先寫,寫完再一起改不就好了?」
這個順序聽起來省事,但實際上把風險留到了最不該留的地方。草稿一旦寫進磁碟,就已經是一份留有痕跡的檔案——即使事後改掉、即使從沒發布,那個版本曾經存在過。如果去識別化只在「發文前」做一次,代表在動筆到掃描之間的這段時間,可識別資訊是以明文形式留在草稿裡的,而不是完全不存在。
去識別化如果只發生在「發文前跑一次 script」,代表寫作過程中大腦是放鬆的——想到什麼案例細節就先寫下來,反正之後會掃。這個做法有兩個問題:一是掃描工具的規則清單不可能涵蓋所有情況(新出現的識別資訊組合,規則清單本來就還沒收錄),二是即使掃描抓到了問題,草稿裡已經明文寫過一次可識別資訊,這個痕跡本身就是風險。
去識別化掃描工具是抓漏網之魚的最後一道防線,不是可以取代動筆當下判斷的替代方案。 已經整理過的素材筆記都曾經漏掉一個真實識別字串沒改——人工複查跟掃描工具都會漏,唯一不會漏的是「一開始就不寫進去」。
回想你上一次寫涉及真實經驗的內容,你是動筆當下就在腦中做了抽象化決定,還是先照實寫、打算事後再回頭改?
Day 09 會用一個真實案例,講一條去識別化規則怎麼從「人工複查漏抓一次」演化成一支自動化掃描工具。
寫這系列文章時,前面幾天也真的在動筆當下抽換過幾個原本想直接寫的具體措辭——這種「寫到一半停下來重新想措辭」的節奏,一開始會覺得打斷思路很煩,但養成習慣之後,反而比事後回頭大改省時間。